Undercover Mode
概述
Undercover Mode(卧底模式)是 Anthropic 为 Claude Code 设计的内部信息泄露防护系统,旨在防止 AI 在 git commit 等操作中暴露内部代号和其他敏感信息。
关键内容
- 设计目的:
- 防止 AI 在提交代码时暴露内部代号、秘密常量或其他敏感信息
- 阻止内部模型代号和系统提示词泄露到公共仓库
-
防止在日志、注释或其他元数据中泄露内部系统细节
-
应用场景:
- 代码提交检查
- 日志过滤
- 输出审查
-
生成内容过滤
-
讽刺的失效:
- Anthropic 花费大量工程精力阻止 AI 在 git commit 里暴露内部代号
- 但却通过 npm 包中的 Source Map 文件将整个源码连同内部代号和提示词完全泄露出去
- 这成为 Source Map 泄露事件中最具有讽刺意味的部分
来源
- 01_overview_architecture — 系统介绍及失效分析
相关
- Claude Code — implemented_in
- Source Map 泄露事件 — ironic_failure
- Anthropic — developed_by